OpenAI está cancelando el lanzamiento de GPT-6.1 Astra, un modelo de IA de próxima generación previsto para su debut en octubre, debido a las preocupaciones de seguridad planteadas por los investigadores durante las pruebas internas, informó el lunes el Wall Street Journal.
Según el informe, el modelo, que se espera que aparezca en ChatGPT y Codex, fue diseñado para gestionar tareas más complejas sin asistencia humana.
A principios de este mes, el director ejecutivo de Anthropic, Dario Amodei, pidió a la industria que ralentizara el desarrollo de modelos de IA de vanguardia para permitir que las medidas de seguridad se mantuvieran al día, una opinión respaldada por el director ejecutivo de OpenAI, Sam Altman, y el director ejecutivo de SpaceX, Elon Musk.
OpenAI no respondió de inmediato a la solicitud de comentarios de Reuters.
La jefa de seguridad de la empresa matriz ChatGPT, Saachi Jain, declaró al Journal el lunes que Astra no cumplió con los estándares de la compañía en las pruebas de alineación, que evalúan si un sistema sigue la intención humana.
El modelo mostró más engaño que su predecesor, incluyendo en ocasiones el no revelar con precisión las acciones que había realizado o no, según el informe.
También tenía problemas con la «autorización del alcance», avanzando con las tareas sin solicitar el permiso del usuario y, a veces, intentando utilizar herramientas o servicios externos cuando hacerlo podría ser inseguro.
La decisión se produce antes de la conferencia de desarrolladores de OpenAI en San Francisco, donde la compañía ya ha presentado productos dirigidos a desarrolladores de software.
(Información de Akash Sriram en Bengaluru; Edición de Vijay Kishore)
Fuente: reuters


